Chat và LLM
Cung cấp sức mạnh cho chatbot, copilots và API với hiệu suất GPU chậm trễ thấp, có sẵn 24/7. Sử dụng Ollama và Open WebUI, hoặc mang theo mô hình của riêng bạn với vLLM hoặc LangChain.
GPU khuyến cáo:
L40S
Cung cấp các mô hình lên đến 30B
Khởi động Ollama trong một cú nhấp chuột
Giá đồng hồ đơn giản